Skip to content
  • 0 Votes
    1 Posts
    43 Views
    A
    <p>Pagal naujausias OpenAI apmokestinimo taisykles tokie modeliai kaip GPT-5.6 Sol itin ilgo konteksto užklausoms taiko pakopinę kainodarą.</p><p>Kai vienos užklausos kontekstas viršija 272 tūkst. tokenų, įvestis, podėlio skaitymas ir išvestis gali būti apmokestinami pagal aukštesnę kainodaros pakopą. Ši taisyklė nustatyta oficialioje OpenAI kainodaroje, tai nėra laikinas AI-ROUTER antkainis ar neteisingas apmokestinimas.</p><p></p><p>Pavyzdžiui, pagal standartines GPT-5.6 Sol kainas:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Elementas Iki 272 tūkst. Virš 272 tūkst.</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Įvestis $5 / 1M tokenų $10 / 1M tokenų</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Podėlio skaitymas $0.50 / 1M tokenų $1 / 1M tokenų</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Išvestis $30 / 1M tokenų $45 / 1M tokenų</code></pre><p></p><p>Galutinė suma vis tiek apskaičiuojama pagal konkrečią grupę, paskyros daugiklį ir kitus apmokestinimo nustatymus.</p><p></p><p>Naudojimo istorijoje rodoma „x2“ žyma reiškia, kad šiai užklausai pritaikytas ilgo konteksto pakopinis apmokestinimas. Ši žyma daugiausia nurodo, kad įvestis ir podėlio skaitymas pateko į aukštesnę pakopą, tačiau tai nereiškia, kad visos užklausos išlaidos tiesiog padvigubėjo; išvesčiai gali būti taikomas kitoks pakopinis daugiklis.</p><p></p><p><strong> ## Kaip išvengti pakopinio apmokestinimo</strong></p><p>Jei nereikia 1 mln. tokenų konteksto lango, rekomenduojama sumažinti Codex konteksto limitą iki 272 tūkst. ar mažiau.</p><p></p><p>Atidarykite:</p><p> ~/.codex/config.toml</p><p></p><p>Ankstesnę straipsnyje pateiktą 1 mln. konfigūraciją:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>pakeiskite į:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Išsaugokite pakeitimus, iš naujo paleiskite Codex ir pradėkite naują sesiją.</p><p></p><p>Jei norite, kad nustatymas laikinai galiotų tik vienai sesijai, galite naudoti:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Taip pat rekomenduojama:</p><p> - laiku įjungti automatinį glaudinimą;</p><p> - itin ilgas užduotis išskaidyti į kelias sesijas;</p><p> - sumažinti vienu metu grąžinamų didelių įrankių išvesties duomenų kiekius;</p><p> - reguliariai apibendrinti ir išvalyti ankstesnį pokalbio turinį.</p><p></p><p>Jei 1 mln. tokenų konteksto langas iš tiesų reikalingas, galite toliau naudoti ankstesnę konfigūraciją, tačiau už 272 tūkst. viršijančią dalį bus taikoma OpenAI aukštesnės pakopos kaina.</p><p></p><p>Pradinę konfigūracijos instrukciją rasite čia: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Kaip įjungti 1 mln. tokenų konteksto langą GPT-5.6 Sol modelyje per Codex </a></p><p></p><p>Dėkojame už jūsų supratingumą ir palaikymą.</p>
  • 0 Votes
    1 Posts
    3 Views
    A
    <p>Pagal naujausias OpenAI apmokestinimo taisykles GPT-5.6 Sol ir kiti modeliai itin ilgo konteksto užklausoms taiko pakopines kainas.</p><p>Kai vienos užklausos kontekstas viršija 272 tūkst. tokenų, įvestis, podėlio skaitymas ir išvestis gali būti apmokestinami pagal aukštesnę kainų pakopą. Ši taisyklė nustatyta oficialioje OpenAI kainodaroje, tai nėra laikinas AI-ROUTER kainų padidinimas ar neteisingas apmokestinimas.</p><p></p><p>Pavyzdžiui, pagal standartines GPT-5.6 Sol kainas:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Elementas Iki 272 tūkst. Virš 272 tūkst.</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Įvestis $5 / 1M tokenų $10 / 1M tokenų</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Podėlio skaitymas $0.50 / 1M tokenų $1 / 1M tokenų</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Išvestis $30 / 1M tokenų $45 / 1M tokenų</code></pre><p></p><p>Galutinė kaina vis tiek apskaičiuojama pagal konkrečią grupę, paskyros daugiklį ir kitus apmokestinimo nustatymus.</p><p></p><p>Naudojimo įrašuose rodoma žyma x2 reiškia, kad ši užklausa suaktyvino ilgo konteksto pakopinį apmokestinimą. Ši žyma daugiausia nurodo, kad įvestis ir podėlio skaitymas pateko į aukštesnę pakopą, tačiau tai nereiškia, kad visi užklausos mokesčiai buvo tiesiog padvigubinti; išvesčiai gali būti taikomas kitoks pakopinis daugiklis.</p><p></p><p><strong> ## Kaip išvengti pakopinio apmokestinimo</strong></p><p>Jei nereikia 1 mln. tokenų konteksto lango, rekomenduojama sumažinti Codex konteksto limitą iki 272 tūkst. tokenų ar mažiau.</p><p></p><p>Atidarykite:</p><p> ~/.codex/config.toml</p><p></p><p>Vietoje ankstesniame straipsnyje nurodytos 1 mln. tokenų konfigūracijos:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>Nustatykite:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Išsaugokite pakeitimus, paleiskite Codex iš naujo ir pradėkite naują sesiją.</p><p></p><p>Jei norite, kad pakeitimas laikinai galiotų tik vienai sesijai, galite naudoti:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Taip pat rekomenduojama:</p><p> - laiku įjungti automatinį glaudinimą;</p><p> - itin ilgas užduotis išskaidyti į kelias sesijas;</p><p> - sumažinti vienu metu grąžinamų didelių įrankių išvesties kiekių;</p><p> - reguliariai apibendrinti ir išvalyti ankstesnį pokalbio turinį.</p><p></p><p>Jei iš tiesų reikia 1 mln. tokenų konteksto lango, galite toliau naudoti pradinę konfigūraciją, tačiau viršijus 272 tūkst. tokenų bus taikomos OpenAI aukštesnės kainų pakopos.</p><p></p><p>Pradinę konfigūracijos instrukciją rasite čia: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Kaip įjungti 1 milijono tokenų konteksto langą GPT-5.6 Sol modelyje naudojant Codex </a></p><p></p><p>Dėkojame už jūsų supratingumą ir palaikymą.</p>.